01. 简介

我们将会应用 Q-learning 算法完成一个经典的 Markov 决策问题 -- 走迷宫!

请查看项目详情 https://github.com/udacity/MLND_CN_P5_Reinforcement_Learning